Skip to content
  • 0 Votes
    1 Posts
    56 Views
    A
    <p>Selon les dernières règles de tarification d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification par paliers aux requêtes utilisant un contexte très long.</p><p>Lorsque le contexte d’une requête dépasse 272K tokens, l’entrée, la lecture du cache et la sortie peuvent être facturées selon des paliers tarifaires supérieurs. Cette règle provient de la tarification officielle d’OpenAI ; il ne s’agit ni d’une majoration temporaire d’AI-ROUTER ni d’une facturation anormale.</p><p></p><p>Exemple avec les tarifs standard de GPT-5.6 Sol :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Élément Jusqu’à 272K Plus de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrée 5 $ / 1M tokens 10 $ / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lecture du cache 0,50 $ / 1M tokens 1 $ / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sortie 30 $ / 1M tokens 45 $ / 1M tokens</code></pre><p></p><p>Le montant final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.</p><p></p><p>La présence du marqueur x2 dans l’historique d’utilisation signifie que la requête a déclenché la tarification par paliers pour contexte long. Ce marqueur indique principalement que l’entrée et/ou la lecture du cache sont passées au palier supérieur ; il ne signifie pas que tous les frais de la requête ont simplement été doublés. La sortie peut être soumise à un multiplicateur de palier différent.</p><p></p><p><strong> ## Comment éviter de déclencher la tarification par paliers</strong></p><p>Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.</p><p></p><p>Ouvrez :</p><p> ~/.codex/config.toml</p><p></p><p>Remplacez la configuration à 1M présentée dans l’article précédent :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>par :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Après l’enregistrement, redémarrez Codex et créez une nouvelle session.</p><p></p><p>Si vous souhaitez appliquer ce réglage temporairement à une seule session, vous pouvez utiliser :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Il est également recommandé de :</p><p> - activer rapidement la compression automatique ;</p><p> - répartir les tâches très longues sur plusieurs sessions ;</p><p> - réduire la quantité de sorties d’outils renvoyées en une seule fois ;</p><p> - résumer et nettoyer régulièrement le contenu plus ancien des conversations.</p><p></p><p>Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine, mais la partie dépassant 272K sera facturée selon les tarifs des paliers supérieurs d’OpenAI.</p><p></p><p>Pour consulter les instructions de configuration d’origine, reportez-vous à : <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol </a></p><p></p><p>Merci de votre compréhension et de votre soutien.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>Selon les dernières règles de facturation d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification progressive aux requêtes utilisant un contexte ultra-long.</p><p>Lorsque le contexte d’une requête dépasse 272K tokens, les tokens d’entrée, de lecture du cache et de sortie peuvent être facturés selon un niveau tarifaire supérieur. Cette règle provient de la tarification officielle d’OpenAI ; il ne s’agit pas d’une majoration temporaire ni d’une facturation anormale d’AI-ROUTER.</p><p></p><p>À titre d’exemple, voici les tarifs standard de GPT-5.6 Sol :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Élément Jusqu’à 272K Au-delà de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrée $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lecture cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sortie $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Le coût final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.</p><p></p><p>La présence du marqueur x2 dans l’historique d’utilisation signifie que la requête a déclenché la tarification progressive du contexte long. Ce marqueur indique principalement que l’entrée et la lecture du cache sont passées au niveau tarifaire supérieur ; il ne signifie pas que tous les frais de la requête ont simplement doublé. La sortie peut être soumise à un multiplicateur différent selon le niveau tarifaire.</p><p></p><p><strong>## Comment éviter de déclencher la tarification progressive</strong></p><p>Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.</p><p></p><p>Ouvrez :</p><p> ~/.codex/config.toml</p><p></p><p>Remplacez la configuration de 1M tokens indiquée dans l’article précédent :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>par :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Enregistrez le fichier, redémarrez Codex et créez une nouvelle session.</p><p></p><p>Pour appliquer temporairement ces paramètres à une seule session, utilisez :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Il est également recommandé de :</p><p> - activer rapidement la compression automatique ;</p><p> - diviser les tâches très longues en plusieurs sessions ;</p><p> - réduire la quantité de sorties d’outils renvoyées en une seule fois ;</p><p> - résumer et nettoyer régulièrement le contenu plus ancien des conversations.</p><p></p><p>Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine, mais les tokens au-delà de 272K seront facturés selon les tarifs élevés des niveaux supérieurs d’OpenAI.</p><p></p><p>Pour consulter les explications relatives à la configuration d’origine, reportez-vous à : <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol </a></p><p></p><p>Merci de votre compréhension et de votre soutien.</p>
  • 0 Votes
    1 Posts
    70 Views
    A
    <p>Selon les dernières règles de tarification d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification progressive aux requêtes utilisant un contexte très long.</p><p>Lorsque le contexte d’une requête unique dépasse 272K tokens, les tokens d’entrée, de lecture du cache et de sortie peuvent être facturés selon un niveau tarifaire supérieur. Cette règle provient de la tarification officielle d’OpenAI et ne correspond ni à une majoration temporaire d’AI-ROUTER ni à une facturation anormale.</p><p></p><p>À titre d’exemple, voici les tarifs standard de GPT-5.6 Sol :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Élément Jusqu’à 272K Au-delà de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrée $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lecture cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sortie $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Le coût final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.</p><p></p><p>La présence du marqueur x2 dans l’historique d’utilisation indique que cette requête a déclenché la tarification progressive applicable aux contextes longs. Ce marqueur signifie principalement que l’entrée et la lecture du cache sont passées à un niveau tarifaire supérieur. Il ne signifie pas que tous les frais de la requête sont simplement multipliés par deux ; la sortie peut être soumise à un multiplicateur différent selon le niveau tarifaire.</p><p></p><p><strong> ## Comment éviter de déclencher la tarification progressive</strong></p><p>Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.</p><p></p><p>Ouvrez :</p><p> ~/.codex/config.toml</p><p></p><p>Remplacez la configuration à 1M tokens présentée dans l’article d’origine :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>par :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Après l’enregistrement, redémarrez Codex et créez une nouvelle session.</p><p></p><p>Si vous souhaitez appliquer ce réglage temporairement à une seule session, vous pouvez utiliser :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Il est également recommandé de :</p><p> - activer rapidement la compression automatique ;</p><p> - répartir les tâches très longues sur plusieurs sessions ;</p><p> - réduire la quantité de sorties d’outils renvoyées en une seule fois ;</p><p> - résumer et nettoyer régulièrement le contenu plus ancien des conversations.</p><p></p><p>Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine. Toutefois, la partie dépassant 272K sera facturée selon les tarifs élevés d’OpenAI correspondant aux niveaux supérieurs.</p><p></p><p>Pour consulter les instructions de configuration d’origine, voir : <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol </a></p><p></p><p>Merci de votre compréhension et de votre soutien.</p>